技術2026年5月14日(木)約29分oMLX 0.3.9.dev2をM1 Max 64GBで実測、SSD KVキャッシュ・Gemma 4 VLM MTP・DFlash・omlx launch copilotM1 Max 64GBにoMLX 0.3.9.dev2を入れて、SSD KVキャッシュ2回目prefill短縮、Gemma 4 VLM MTPオン/オフ、DFlash vs 通常エンジン、omlx launch copilotの実動作を順に測る。VLM入力はWAI-Animaで生成したかなちゃん画像で揃えた。AILLMローカルLLMApple SiliconMLX推論最適化Codex実験
技術2026年5月13日(水)約7分Quake IIIの高速逆平方根(0x5f3759df)をApple M4とZen 3で実機ベンチ、std::sqrtより速くなる条件がプラットフォームで違ったApple M4 (Mac mini) と Zen 3 (Ryzen 5800HS / WSL2) でFISRを実機ベンチ。M4は-O2で1/sqrtfがrsqrte化されQ_rsqrtに肉薄、Zen 3は-ffast-math必須で-O2のままだと12倍差。自前NEON/SSEは逆に遅い、ニュートン回数別の誤差、Lomont定数比較も込み。CアルゴリズムベンチマークApple Silicon数学ゲーム開発実験
技術2026年5月13日(水)更新約7分oMLX 0.3.9.dev2はMacローカルLLMをCodexやCopilotに寄せてきたoMLX 0.3.9.dev2のリリースノートを読む。Gemma 4 VLMのMTP、DFlash対応、SSD KVキャッシュ、`omlx launch copilot`まわりが、Codex/Copilotなど常駐エージェントをMacローカルLLMに繋ぐ時にどこへ効くかを整理した。AILLMローカルLLMApple SiliconMLX推論最適化Codex
技術2026年5月8日(金)約10分FLUX.2 Klein 9B + 9B NSFW LoRAをM1 Max 64GB / mflux 0.17.5で実機検証するM1 Max 64GBでFLUX.2 Klein 9B + diroverflo/FLux_Klein_9B_NSFWを実際に動かした記録。NSFWプロンプトで実際にNSFW画像が出ることまで確認。4bit量子化で512は1分51秒、1024は5分37秒、LoRAのオーバーヘッドはほぼゼロAI画像生成FLUXApple SiliconMacMLXLoRA実験
技術2026年5月4日(月)更新約14分FLUX.2 Kleinの成人向けLoRAはM1 Max環境でそのまま試せるのかFLUX.2 Klein 9B向けの成人向けLoRAをM1 Max 64GBで試せるか調べた。モデル互換性、LoRA適用経路、RunPod検証に加え、自前でLoRA学習する場合のVRAM要件やai-toolkitの設定も整理した。AI画像生成FLUXApple SiliconMacMLXLoRA実験
技術2026年5月3日(日)約9分日本語プロンプトをOllamaで英訳してComfyUIとmfluxに投げるFastAPIラッパでAnima・WAI-IL・FLUX.2 KleinをまとめてWebUI化ローカルにあるWAI-Anima・WAI-IL(SDXL)・FLUX.2 Klein 4Bの3エンジンを、日本語プロンプトのまま叩ける薄いFastAPIラッパで束ねる。翻訳はOllama (gemma3:12b)、ComfyUIはAPIで動的にワークフロー組み立て、FLUX.2はmflux CLIをsubprocess、Tailscale経由でiPhoneからも生成できるようにした。AI画像生成ComfyUIFLUXApple SiliconMacOllamaFastAPITailscale実験
技術2026年5月2日(土)約22分FastAPI・Chroma・Open WebUI・Ollamaでマルチモーダル日本語RAGをM1 Maxで組んだDEV記事のPDF RAGをM1 Max 64GBで実装し、CLIPで画像、bge-m3 + Qwen3.6 35Bで日本語まで通した実験ログ。モダリティギャップ、推論サーバー並走クラッシュ、LLM-jp 4-8Bの指示追従失敗まで実機の挙動を記録。AILLMRAGローカルLLMFastAPIllama.cppChromaPythonApple SiliconOllama日本語LLM実験
技術2026年5月2日(土)約19分Qwen-ScopeのSAEをM1 Max 64GBで動かして日本語特徴を取り出すQwen-ScopeのSparse AutoencoderをローカルのM1 Max 64GBで動かし、Qwen3-8B-Baseの中間層から日本語・英語・コード・中国語を弁別する特徴IDを取り出した記録。AILLMQwen解釈可能性実験Apple SiliconMPS
技術2026年4月30日(木)更新約11分mflux vs iris.cでFLUX.2 Klein 4Bを動かしたM1 MaxベンチFLUX.2 Klein 4BをM1 Max 64GB上で、mflux(MLX)とiris.c(純C+Metal)の2系統で実機ベンチ。Pruna AIのH100前提チュートリアルへのカウンターとして、Apple Siliconで何秒で出るかを実測した。AI画像生成FLUXApple SiliconMacMLX実験
技術2026年4月30日(木)約8分Xiaomi MiMo-V2.5はMacやROCmで動かせるのかXiaomi MiMo-V2.5のウェイト公開後、Mac/ROCmとクラウドGPU(RunPod/GCE)での実行可否を調べた。手元機ではまだ厳しいが、RunPodの4x H200で約14ドル/時間、GCE SpotのH100なら約1.6ドル/時間で動かせる。AILLMローカルLLMXiaomiMoEApple SiliconROCmllama.cpp
技術2026年4月29日(水)更新約13分Z-AnimeはZ-Image系のアニメ特化フルファインチューンだったSeeSee21/Z-AnimeがZ-Image Baseのフルファインチューンであることを確認し、AIO版をM1 Max 64GBのローカルComfyUIで動かしてt2i・i2i・NSFW通り具合まで検証した。AI画像生成Z-ImageComfyUIApple Silicon実験
技術2026年4月29日(水)約14分AIイラストを漫画モノクロに変換するときグレスケではなくスクリーントーンにしたい話カラーのアニメ系AIイラストを漫画原稿風のモノクロへ変換する検証ログ。AI再生成系は色残りか顔変化のどちらかに寄り、決定論的なローカル処理だけだと機械的に見える。次に試すべき方向(Anima にグレスケ専用LoRAを載せる案、See-throughで部位分離してから機械合成する案)まで整理する。AI画像生成ComfyUILoRA漫画スクリーントーン実験Apple SiliconSDXLQwenZ-ImageAnima